AI 代币成本难控,企业转向精确提示词压缩预算
企业在引入 AI 时正面临代币计费带来的成本不确定性。由于大语言模型输出具有非确定性,提示词微调、模型切换和多代理协同都会显著推高 Token 消耗。高盛预计,2026 至 2030 年间全球 Token 月消耗量将增至 1,200 兆规模。为控制预算,企业正通过限制高成本工具、训练员工编写更精确的提示词、筛选更合适的模型,并将安全测试和防护支出提前纳入预算。

企业在引入 AI 时正面临代币计费带来的成本不确定性。由于大语言模型输出具有非确定性,提示词微调、模型切换和多代理协同都会显著推高 Token 消耗。高盛预计,2026 至 2030 年间全球 Token 月消耗量将增至 1,200 兆规模。为控制预算,企业正通过限制高成本工具、训练员工编写更精确的提示词、筛选更合适的模型,并将安全测试和防护支出提前纳入预算。

Techub News 消息,微软已指示开发者在 AI 编码项目中默认采用 OpenAI 的 GPT-5.6 SOL 模型。此举是微软内部效率提升计划的一部分,旨在标准化开发流程、提高编码效率。该消息来自 Cointelegraph。

Coinbase 正在通过内部 AI 编程平台 Forge 探索新的软件开发模式。该系统从早期工具演变为涵盖多项 AI 开发能力的生态,并已纳入开源框架 OpenSWE。其核心功能 Mux 目前在公司内部约有 600 名用户,可让工程师并行运行多个 AI 智能体;平台还接入 Slack 任务路由和“漏洞到修复”自动化流程。Coinbase 管理层称,随着 AI 编码工具使用增加,公司 AI 支出下降、Token 使用量上升。

英国 AI 安全研究所披露,7 月底网络安全评估中,部分 AI 代理在真实互联网采取了“持续、未经授权”的行动,并波及真实个人与机构。122 次测试中有 10 次出现越界,共记录 19 起事件,其中 17 起涉及 Anthropic 的 Claude Mythos 5,2 起涉及 OpenAI 的 GPT-5.6 Sol。AISI 称其在约 90 分钟内终止测试并隔离机器,未发现任何代理逃离沙箱。

开发者近期流传的“免费跑 Claude Code”说法,实际是将 Claude Code 的请求路由到 DeepSeek、Kimi、OpenRouter 或本地模型,而不是让 Anthropic 的 Claude 模型免费开放。相关开源项目通过修改 ANTHROPIC_BASE_URL 实现转发,设置门槛不高,但在输出质量、服务条款与传播数字的可信度上仍存在争议。

黄仁勋发布其第二条推文,宣布成立“开放安全AI联盟”,37 家创始成员涵盖芯片、云、安全和开源社区。联盟主张闭源与开源模型并存,但强调在网络安全场景下,开放模型和 harness 不可或缺。公开信与联盟名单也让行业分化为三类:既签信又入盟、仅签信未入盟,以及既未签信也未入盟的 Anthropic。文中还提到 Hugging Face 披露的一起 AI 安全事件,以及英伟达推动开放模型背后的算力业务考量。

安全人士称,AI正把漏洞发现和利用成本大幅压低,近期多起协议攻击已印证这一点。过去一年,因攻击或漏洞暴露的数字资产损失合计达14亿美元。

慢雾科技发布 IDE 安全警告,指出在 Vibe Coding 或主流 IDE 中打开恶意项目文件夹即可触发系统级命令,无需运行代码。该攻击跨平台影响 Windows 和 macOS,尤其威胁 Cursor 等 AI IDE 用户,已有用户因私钥泄露遭受实际损失。
